<p>Selon les dernières règles de facturation d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification progressive aux requêtes utilisant un contexte ultra-long.</p><p>Lorsque le contexte d’une requête dépasse 272K tokens, les tokens d’entrée, de lecture du cache et de sortie peuvent être facturés selon un niveau tarifaire supérieur. Cette règle provient de la tarification officielle d’OpenAI ; il ne s’agit pas d’une majoration temporaire ni d’une facturation anormale d’AI-ROUTER.</p><p></p><p>À titre d’exemple, voici les tarifs standard de GPT-5.6 Sol :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Élément Jusqu’à 272K Au-delà de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrée $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lecture cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sortie $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Le coût final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.</p><p></p><p>La présence du marqueur x2 dans l’historique d’utilisation signifie que la requête a déclenché la tarification progressive du contexte long. Ce marqueur indique principalement que l’entrée et la lecture du cache sont passées au niveau tarifaire supérieur ; il ne signifie pas que tous les frais de la requête ont simplement doublé. La sortie peut être soumise à un multiplicateur différent selon le niveau tarifaire.</p><p></p><p><strong>## Comment éviter de déclencher la tarification progressive</strong></p><p>Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.</p><p></p><p>Ouvrez :</p><p> ~/.codex/config.toml</p><p></p><p>Remplacez la configuration de 1M tokens indiquée dans l’article précédent :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>par :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Enregistrez le fichier, redémarrez Codex et créez une nouvelle session.</p><p></p><p>Pour appliquer temporairement ces paramètres à une seule session, utilisez :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Il est également recommandé de :</p><p> - activer rapidement la compression automatique ;</p><p> - diviser les tâches très longues en plusieurs sessions ;</p><p> - réduire la quantité de sorties d’outils renvoyées en une seule fois ;</p><p> - résumer et nettoyer régulièrement le contenu plus ancien des conversations.</p><p></p><p>Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine, mais les tokens au-delà de 272K seront facturés selon les tarifs élevés des niveaux supérieurs d’OpenAI.</p><p></p><p>Pour consulter les explications relatives à la configuration d’origine, reportez-vous à : <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol </a></p><p></p><p>Merci de votre compréhension et de votre soutien.</p>